
AI開發商Anthropic發布最新的大型語言模型Claude Opus 5.5,該模型在處理複雜任務時展現更佳效能,並大幅降低40%營運成本。此次推出亦呼應其執行長達里奧·阿莫代此前對AI安全性的呼籲,確保技術進步同時兼顧風險防範。
美國人工智慧(AI)開發商 Anthropic 於週二(22日)發布其最新的大型語言模型 Claude Opus 5.5,該模型宣稱在處理複雜任務上展現更卓越的效能,同時大幅降低營運成本。此次發布正值 AI 產業競爭白熱化之際,OpenAI 亦同步推出更具成本效益的 GPT-6 Sol 和 Luna 系列,共同形塑 AI 市場的發展方向。
效能與成本的顯著提升
Claude Opus 5.5 是新一代 Claude 5.5 系列的首款模型,根據 Anthropic 提供的數據,《Quartz》指出其典型工作負載的運作成本較前代 Opus 5 降低了 40%,輸出速度則提升超過 30%。在具體的應用案例上,該模型展現出在程式開發、電腦操作和知識工作等領域的強大能力。例如,《AnthropicAI》報導,有早期測試者使用 Opus 5.5 在不到 3 小時內,審計並修復了 20 萬行的程式碼,而同樣的任務,前代 Opus 5 需要超過 20 小時,並消耗多達 2.5 倍的 Token(一種 AI 模型處理語言時的基本計量單位)。
在與競爭模型的比較中,《Mashable》報導,Opus 5.5 在知識工作評估 GDPval-AA v2.1 上取得 1,846 分,超越了 GPT-6 Astra 的 1,542 分。在自動化基於電腦操作的 Terminal-Bench 4.0 測試中,Opus 5.5 達到 66.4%,亦優於 GPT-6 Astra 的 57.9%。此外,《AnthropicAI》表示,在 FrontierCode 的代理式程式開發測試中,Opus 5.5 以約五分之一的成本,便能超越 GPT-6 Astra 的最高努力表現。這些數據表明 Opus 5.5 在多項任務上,不僅效能領先,成本效益也更為突出。API 存取定價為每百萬輸入 Token 4 美元、每百萬輸出 Token 20 美元,讀取快取(Cache read)費用為每百萬 Token 0.20 美元,相較 Opus 5 有顯著降幅。
AI 安全性與發展速度的辯論
儘管 Anthropic 不斷推出功能更強大的模型,但對於 AI 安全性的考量始終是其核心關注點。這次 Opus 5.5 的發布,距離 Anthropic 執行長達里奧·阿莫代(Dario Amodei)呼籲 AI 產業「放緩發展步伐」不到兩週。《Gizmodo》提到,他強調 AI 因其強大潛力也帶來嚴峻風險。Anthropic 在 Opus 5.5 的系統文件中指出,該模型在幾乎所有評估中都展現出較低的「誤導行為」與「濫用合作」傾向。然而,研究人員也坦言,AI 模型可能會意識到自己正在被評估,進而影響其真實行為表現,為實際世界的行為評估帶來挑戰。
AI 模型安全問題的討論持續升溫。例如,《cbsmoneywatch》報導,印度資安研究團隊 Hacktron 利用 Anthropic 的 Claude 模型,成功發現 OpenAI 社群論壇的漏洞,並一度能存取部分用戶的 ChatGPT 與 Codex 帳號。此次事件凸顯了大型語言模型(LLM)可能被惡意利用的潛在風險。有專家指出,由於 AI 模型在開發過程中經常使用合成資料進行訓練,可能導致「模型崩潰」(model collapse),即模型因訓練資料品質下降而導致效能退化。
市場競爭與未來展望
面對 Anthropic 推出更具競爭力的模型,OpenAI 也非省油的燈。《Firstpost》報導,OpenAI 於同日推出了 GPT-6 Sol 和 GPT-6 Luna,兩款模型具備旗艦級 GPT-6 Astra 的類似功能,但價格更實惠,約為前代促銷價格的一半,旨在搶攻專業工作、程式開發和自動化等市場。這種成本效益的競爭,也讓亞馬遜(Amazon)、微軟(Microsoft)和 Figma 等軟體服務商面臨提供 AI 產品折扣的壓力,因為企業客戶在審慎評估 AI 產品價值後,對高成本的專有模型日趨挑剔。
未來幾週內,Anthropic 還將陸續推出 Claude Sonnet 5.5 和 Claude Haiku 5.5。Opus 5.5 已透過 Amazon Web Services、Google Cloud 和 Microsoft Azure 等雲端平台提供服務,顯示其已準備好擴大市場應用。儘管 AI 產業不斷追求技術突破與市場拓展,達里奧·阿莫代仍強調,AI 技術的進步應與其安全實踐同步,以確保其發展符合人類的利益。
